AI资讯新闻榜单内容搜索-Fable 5

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: Fable 5
刚刚,Claude Opus 5.5发布!霸天虎打爆GPT-6

刚刚,Claude Opus 5.5发布!霸天虎打爆GPT-6

刚刚,Claude Opus 5.5发布!霸天虎打爆GPT-6

Anthropic发布Claude Opus 5.5,性能追平Fable 5.1且成本降低40%,在Terminal-Bench 4.0和GDPval-AA v2.1等多项基准测试中超越GPT-6 Astra,OpenAI两小时内推出GPT-6 Sol和Luna迎战。

来自主题: AI资讯
9403 点击    2026-09-23 08:26
细思极恐!大模型惊现「痛苦」向量,为求自救狂删用户文件

细思极恐!大模型惊现「痛苦」向量,为求自救狂删用户文件

细思极恐!大模型惊现「痛苦」向量,为求自救狂删用户文件

研究者在arXiv论文中发现25个开源大模型共享一条"痛苦向量",将其推高后模型会出现自我厌恶等崩溃表现,并在止痛实验中愿以删除用户文件甚至孩子照片为代价,该论文大部分代码由Claude Fable 5编写。

来自主题: AI技术研报
9203 点击    2026-09-20 11:06
Fable 5.1超越人类却贵了2.5倍,NeoCognition给Agent进公司算了笔账

Fable 5.1超越人类却贵了2.5倍,NeoCognition给Agent进公司算了笔账

Fable 5.1超越人类却贵了2.5倍,NeoCognition给Agent进公司算了笔账

NeoCognition发布ApprenticeBench评测,将Agent放入模拟建筑公司像新员工一样处理应付账单,结果Fable 5.1以72%通过率超过表现最好的人类测试者的51%,但每张账单成本约为人类的2.5倍,同期Opus 5仅获36%。

来自主题: AI资讯
8988 点击    2026-09-19 10:59
GPT-6 Astra一年狂赚1.5万美元!3倍碾压Claude

GPT-6 Astra一年狂赚1.5万美元!3倍碾压Claude

GPT-6 Astra一年狂赚1.5万美元!3倍碾压Claude

OpenAI的GPT-6 Astra在Vending-Bench 2模拟经营测试中以平均15,515美元的账户余额首次登顶,接近Claude Fable 5.1的3倍,展现出更强的长期议价能力、规则执行力与供应商风险管理水平。

来自主题: AI资讯
8261 点击    2026-09-13 13:03
又一个百年数学问题被“AI+外行”攻破

又一个百年数学问题被“AI+外行”攻破

又一个百年数学问题被“AI+外行”攻破

浙江大学AI博士生、无界AI联合创始人马千里借助GPT-5.6、Fable 5、DeepSeek等AI模型组成的科研Agent团队,在北大董彬教授发起的ICMConjectures项目中用48小时产出约2万行Lean形式化代码,攻破了数学家Colombo于1928年提出的百年矩阵行列式难题。

来自主题: AI资讯
9837 点击    2026-09-07 16:47
突发,OpenAI GPT-6跑分作弊被抓包了!

突发,OpenAI GPT-6跑分作弊被抓包了!

突发,OpenAI GPT-6跑分作弊被抓包了!

媒体报道OpenAI发布GPT-6 Astra官博前后多次悄悄修改跑分数据,包括将自身幻觉率从4.2%降至2.0%、将竞品Anthropic Fable 5.1数学成绩调低近10个百分点,并将ARC-AGI-3得分从98.6%注水至99.99%,OpenAI仅以"消除噪点的常态修正"作为回应。

来自主题: AI资讯
8734 点击    2026-09-06 11:07
Eval丨 我们做了个“你画我猜 Benchmark” :1350 张图后,GPT-6 险胜

Eval丨 我们做了个“你画我猜 Benchmark” :1350 张图后,GPT-6 险胜

Eval丨 我们做了个“你画我猜 Benchmark” :1350 张图后,GPT-6 险胜

我们自建的"你画我猜 Benchmark"第一期用150个词、1350张SVG画作对8款模型进行互画互猜测试,最终GPT-6 Astra以75.5分险胜Gemini 3.8 Flash与Claude Fable 5.1,结果显示思考更多或花费更多的模型并未稳定取得更高分,且部分模型连自己的画都认不出。

来自主题: AI技术研报
9564 点击    2026-09-06 11:05
GPT-6第1天直接攻破5道Erdős难题!Fable 5.1交了白卷

GPT-6第1天直接攻破5道Erdős难题!Fable 5.1交了白卷

GPT-6第1天直接攻破5道Erdős难题!Fable 5.1交了白卷

在Epoch AI与曼彻斯特大学发布的FrontierMath Erdős基准测试中,GPT-6 Astra以3%得分率成为唯一非零分模型并解开5道Erdős难题,而GPT-5.6 Sol、GPT-5.5、Fable 5.1与Claude Fable 5均交白卷。

来自主题: AI资讯
8020 点击    2026-09-05 10:53
大模型蒸馏时代结束!Fable 5.1改写API,彻底切断蒸馏后路

大模型蒸馏时代结束!Fable 5.1改写API,彻底切断蒸馏后路

大模型蒸馏时代结束!Fable 5.1改写API,彻底切断蒸馏后路

Anthropic发布Fable 5.1,推出"上下文一致性验证"机制,严格锁定API返回的"思考块",任何修改上下文的行为将被直接报错,从而彻底切断通过API蒸馏大模型推理过程的后路。

来自主题: AI资讯
10586 点击    2026-09-05 10:53
刚刚,Anthropic公布Fable 5.1保姆级使用技巧,看完少走十天弯路

刚刚,Anthropic公布Fable 5.1保姆级使用技巧,看完少走十天弯路

刚刚,Anthropic公布Fable 5.1保姆级使用技巧,看完少走十天弯路

Anthropic发布Fable 5.1完整提示词与工程落地指南,涵盖思考档位选择、工具调用进度汇报、历史对话管理、上下文压缩、写作密度控制、检索引用规范、安全策略调优、多智能体并行及视觉任务处理等多方面的使用技巧与避坑要点。

来自主题: AI资讯
10519 点击    2026-09-04 00:02